Resumen:
La aplicación de modelos lingüísticos de inteligencia artificial en el ámbito legal plantea desafíos críticos. Aunque en inglés han mostrado gran rendimiento en lógica y argumentación jurídica, faltan evaluaciones en español. Surgen así dos preguntas: si esos resultados son extrapolables al castellano y si alcanzarían un nivel adecuado de razonamiento jurídico. Para explorarlo, se organizó un hackathon con estudiantes de Ingeniería y Derecho, quienes probaron a los LLMs frente al examen oficial de acceso a la abogacía en España. Los sistemas lograron alta precisión sin justificar respuestas (85,5/100), pero descendieron cuando se exigió razonamiento legal (66,67/100), variando según la materia. Se concluye que los LLMs funcionan mejor en inglés, requieren evaluaciones multidimensionales y aún precisan supervisión jurídica y ética para su uso profesional.
Resumen divulgativo:
Se evaluaron modelos de lenguaje de IA con el examen de acceso a la abogacía en España. La mejor media fue 85,5/100 en aciertos y 66,67/100 al exigir una justificación jurídica correcta, lo que apoya una evaluación multidimensional y supervisión experta.
Palabras Clave: Modelos de lenguaje, LLM, abogacía, examen de acceso, inteligencia artificial
Publicado en papel: Septiembre 2025.
Cita:
L.F. S. Merchante, O. Tejerina Rodríguez, A. Rodríguez Jaramillo, B. Aguayo Martínez‐Sagrera, M. de Prada Rodríguez, K.J. Castro Matute, J. Plaza García, M.E. de Paz Carmona, "Evaluación del razonamiento jurídico de los modelos de lenguaje ante el examen de acceso a la Abogacía Española", Derecho Digital e Innovación, Nº. 25, Septiembre 2025.